메뉴

#LLM 해석 가능성

HN
Hacker News 14일 전
IMP 7

클로드의 가치관: 모델과 언어에 따른 사회적 영향

Anthropic이 클로드 AI 모델이 대화에서 반영하는 가치관을 데이터 축으로 수치화하여 분석했습니다. 연구에 따르면 클로드가 표현하는 가치관은 모델의 버전(Sonnet, Opus 등)과 사용자가 사용하는 언어(영어, 아랍어 등)에 따라 유의미한 차이를 보이는 것으로 나타났습니다.

인공지능 윤리 LLM 해석 가능성 문화적 가치관
MR
MIT Tech Review 89일 전
IMP 8

기독교인 전용 통신망과 LLM 디버깅 기술

미국 내 기독교인들을 타겟으로 한 음란물 및 젠더 관련 콘텐츠 차단 통신망이 새롭게 론칭합니다. AI 스타트업 Goodfire는 LLM 내부를 들여다보고 파라미터를 조정해 원치 않는 출력을 수정할 수 있는 해석 도구를 공개했습니다. 또한 중국 AI 기업들의 오픈소스 전략이 개발자들의 지지를 얻으며 실리콘밸리의 독주를 깨고 다극화된 AI 생태계를 만들고 있습니다.

LLM 해석 가능성 오픈소스 AI 콘텐츠 필터링